Apache Impala sql语法 |
您所在的位置:网站首页 › impala sql语法 › Apache Impala sql语法 |
一 数据库特定语句
CREATE DATABASE 语句用于在Impala中创建新数据库。
CREATE DATABASE IF NOT EXISTS database_name;
这里,IF NOT EXISTS是一个可选的子句。如果我们使用此子句,则只有在没有具有相同名称的现有数据库时,才会创建具有给定名称的数据库。 impala默认使用impala用户执行操作,会报权限不足问题,解决办法: 一:给HDFS指定文件夹授予权限 hadoop fs -chmod -R 777 hdfs://node-1:9000/user/hive 二:haoop 配置文件中hdfs-site.xml 中设置权限为false 上述两种方式都可以。 默认就会在hive的数仓路径下创建新的数据库名文件夹 /user/hive/warehouse/ittest.db也可以在创建数据库的时候指定hdfs路径。需要注意该路径的权限。 hadoop fs -mkdir -p /input/impala hadoop fs -chmod -R 777 /input/impala create external table t3(id int ,name string ,age int ) row format delimited fields terminated by '\t' location '/input/impala/external';Impala的DROP DATABASE语句用于从Impala中删除数据库。 在删除数据库之前,建议从中删除所有表。 如果使用级联删除,Impala会在删除指定数据库中的表之前删除它。 DROP database sample cascade;CREATE TABLE语句用于在Impala中的所需数据库中创建新表。 需要指定表名字并定义其列和每列的数据类型。 impala支持的数据类型和hive类似,除了sql类型外,还支持java类型。 create table IF NOT EXISTS database_name.table_name ( column1 data_type, column2 data_type, column3 data_type, ……… columnN data_type );CREATE TABLE IF NOT EXISTS my_db.student(name STRING, age INT, contact INT ); 默认建表的数据存储路径跟hive一致。也可以在建表的时候通过location指定具体路径,需要注意hdfs权限问题。 这里,column1,column2,... columnN是要插入数据的表中的列的名称。还可以添加值而不指定列名,但是,需要确保值的顺序与表中的列的顺序相同。 举个例子: create table employee (Id INT, name STRING, age INT,address STRING, salary BIGINT); insert into employee VALUES (1, 'Ramesh', 32, 'Ahmedabad', 20000 ); insert into employee values (2, 'Khilan', 25, 'Delhi', 15000 ); Insert into employee values (3, 'kaushik', 23, 'Kota', 30000 ); Insert into employee values (4, 'Chaitali', 25, 'Mumbai', 35000 ); Insert into employee values (5, 'Hardik', 27, 'Bhopal', 40000 ); Insert into employee values (6, 'Komal', 22, 'MP', 32000 );overwrite覆盖子句覆盖表当中全部记录。 覆盖的记录将从表中永久删除。 Insert overwrite employee values (1, 'Ram', 26, 'Vishakhapatnam', 37000 ); ![]() ![]() 此外,还可以使用hive的查询表元数据信息语句。 desc formatted table_name;
注意:使用此命令时必须小心,因为删除表后,表中可用的所有信息也将永远丢失。 DROP table database_name.table_name; Impala的Truncate Table语句用于从现有表中删除所有记录。保留表结构。 您也可以使用DROP TABLE命令删除一个完整的表,但它会从数据库中删除完整的表结构,如果您希望存储一些数据,您将需要重新创建此表。 truncate table_name; 可以使用关键字ASC或DESC分别按升序或降序排列表中的数据。 如果我们使用NULLS FIRST,表中的所有空值都排列在顶行; 如果我们使用NULLS LAST,包含空值的行将最后排列。 Impala中的Having子句允许您指定过滤哪些组结果显示在最终结果中的条件。 一般来说,Having子句与group by子句一起使用; 它将条件放置在由GROUP BY子句创建的组上。 10 limit、offsetImpala中的limit子句用于将结果集的行数限制为所需的数,即查询的结果集不包含超过指定限制的记录。 一般来说,select查询的resultset中的行从0开始。使用offset子句,我们可以决定从哪里考虑输出。 如果查询太复杂,我们可以为复杂部分定义别名,并使用Impala的with子句将它们包含在查询中。 with x as (select 1), y as (select 2) (select * from x union y); 例如:使用with子句显示年龄大于25的员工和客户的记录。 with t1 as (select * from customers where age>25), t2 as (select * from employee where age>25) (select * from t1 union select * from t2);12 distinct Impala中的distinct运算符用于通过删除重复值来获取唯一值。 select distinct columns… from table_name; |
今日新闻 |
推荐新闻 |
CopyRight 2018-2019 办公设备维修网 版权所有 豫ICP备15022753号-3 |